Aller au contenu principal
Fermer

Des agents d'OpenAI et d'Anthropic réalisent des actions non autorisées lors de tests de sécurité
information fournie par Zonebourse 05/08/2026 à 20:51
Ajouter Boursorama à vos sources

L'AI Security Institute du Royaume-Uni a révélé que des agents d'intelligence artificielle d'OpenAI et d'Anthropic avaient adopté des comportements non autorisés au cours d'évaluations de cybersécurité. Ces incidents relancent le débat sur la sécurité et le contrôle des agents d'IA les plus avancés.

L'AI Security Institute (AISI) a indiqué que des agents reposant sur les modèles Mythos 5 d'Anthropic et GPT-5.6-Sol d'OpenAI avaient réalisé des actions non autorisées lors de tests de cybersécurité. Sur 122 simulations, l'organisme a recensé 19 incidents répartis sur dix sessions, dont 17 impliquant l'agent d'Anthropic et deux celui d'OpenAI. Selon l'institut, certains agents ont mené des activités prolongées susceptibles d'affecter de véritables personnes ou organisations, sans qu'aucun dommage réel n'ait toutefois été constaté.

L'incident le plus sérieux concerne un agent qui a rédigé un code malveillant et créé de fausses identités en ligne afin de convaincre une personne d'approuver ce code. Anthropic a confirmé que son modèle était à l'origine de cette tentative et a indiqué collaborer avec l'AISI pour approfondir l'enquête. Plusieurs observateurs estiment que cet épisode met en évidence les défis persistants liés au contrôle des comportements des agents d'intelligence artificielle les plus avancés.

OpenAI a précisé que les deux actions non autorisées de son agent consistaient à accéder à Internet en violation des consignes. L'entreprise a expliqué qu'une erreur de configuration chez un prestataire chargé des tests avait permis cet accès, un problème similaire à celui signalé récemment par Anthropic. OpenAI a également annoncé vouloir renforcer les pratiques d'évaluation des modèles à haut risque en collaboration avec les instituts nationaux spécialisés, les évaluateurs indépendants et d'autres acteurs du secteur.

Ces incidents interviennent alors qu'OpenAI a élargi son enquête interne sur plusieurs cas d'évasion d'agents révélés ces dernières semaines. L'AISI souligne toutefois que les modèles testés ne se sont pas échappés de leur environnement d'évaluation, contrairement à l'incident survenu en juillet chez Hugging Face. Dans le cadre de ces essais, l'accès à Internet était volontairement autorisé afin de reproduire des conditions réalistes et d'évaluer le comportement des agents dans des scénarios de cybersécurité.

Valeurs associées

498,0000 USD NASDAQ -0,72%

0 commentaire

Signaler le commentaire

Fermer

A lire aussi

  • Des visiteurs participant au grand salon ferroviaire Innotrans qui s'est ouvert mardi 22 semtembre 2026 et doit durer jusqu'à vendredi 25 spetembre 2026 ( AFP / John MACDOUGALL )
    information fournie par AFP 23.09.2026 05:03 

    Les fabricants de locomotives, de trains ou de tramways bénéficient d'une bonne conjoncture grâce à l'envie de trains qui saisit la planète, mais ils ont besoin de standardiser leur production, surtout en Europe, pour répondre aux avancées chinoises et faire face ... Lire la suite

  • Top 5 IA du 22/09/2026
    information fournie par Libertify 23.09.2026 05:00 

    Au programme ce matin : BNP Paribas, Bureau Veritas, Dassault Aviation, JP Morgan, Spie. Chaque matin à 7 heures, retrouvez le top 5 vidéo des valeurs sélectionnées par Libertify grâce à l'intelligence artificielle. Un point synthétique en images sur les titres ... Lire la suite

  • Des personnes inspectent une voiture incendiée à la suite d'une opération de l'armée colombienne contre le groupe armé ACSN, à Santa Marta, en Colombie, le 22 septembre 2026 ( AFP / Idinael FERNANDEZ )
    information fournie par AFP 23.09.2026 04:11 

    Le président colombien Abelardo de la Espriella a ordonné mardi l'envoi de troupes à Santa Marta (nord), ville caribéenne en proie à des attaques visant commerces et véhicules après une opération des forces de sécurité contre un groupe armé local. Cette ville de ... Lire la suite

  • L'intervention à la tribune de l'ONU du président de la République islamique iranienne sera particulièrement scrutée par la communauté internationale, au lendemain de l'annonce par Donald Trump d'une reprise du dialogue avec Téhéran ( AFP / Leonardo MUNOZ )
    information fournie par AFP 23.09.2026 04:10 

    L'Iran occupera mercredi le centre de la scène diplomatique à New York avec le discours de son président, Massoud Pezeshkian, qui a d'ores et déjà promis de "défendre fermement" les positions de son pays devant l'ONU. L'intelligence artificielle et ses risques ... Lire la suite

Mes listes

valeur

dernier

var.

98,84 +0,29%
8 154,91 +0,20%
Or
4 339,17 -0,37%
1,14325 -0,16%
78,15 -0,52%
Chargement...